AI 推理服务的 Huge Pages 工程实战——从 THP 陷阱到 PMD 大页调优与 KSM 协同 深入剖析 Linux Transparent Huge Pages 在 AI 推理服务中的尾延迟陷阱,从 TLB Miss 根源出发,详解 khugepaged 工作机制、四种 defrag 策略、GPU 显存映射冲突,并提供静态 hugetlbfs + madvise 精准标记的生产级调优方案。含 BPF 追踪脚本与决策树。 全栈开发 2026年09月30日 0 点赞 0 评论 41 浏览
深入剖析 x86-64 页表与 TLB 管理:从四级页表遍历到虚拟化 EPT/NPT 从硬件机制深入剖析 x86-64 架构的页表与 TLB 管理全貌,涵盖四级页表遍历、TLB 硬件结构、ASID/PCID/VPID、TLB Shootdown 跨核广播、大页对 TLB 的优化、虚拟化 EPT/NPT 双重翻译、Meltdown KPTI 缓解,以及生产环境中的 perf 调优实战与配置最佳实践。 云计算 2026年09月30日 0 点赞 0 评论 45 浏览
从 x86-64 四级页表到 ARM64 五级页表:Linux 内核页表遍历在 AI 推理大内存场景中的深度工程 深入剖析 Linux 内核页表遍历机制如何成为 AI 推理性能的关键瓶颈,涵盖 x86-64 四级/五级页表、ARM64 LPA2 扩展、Huge Pages 策略、TLB 优化、NUMA 本地化以及 CXL 内存分层实战。 内存管理 2026年10月07日 0 点赞 0 评论 28 浏览